Type: concept
Confidence: 0.90
Created: 2026-04-20
Updated: 2026-04-25
Tags: generative modelstext-to-imagediffusion models深度学习

Stable Diffusion

概述

Stable Diffusion是一种基于潜在空间的扩散模型,用于高质量文本到图像生成,具有高效性和可控性。

关键内容

  1. 潜在扩散模型:在预训练的自动编码器的潜在空间中执行扩散过程,大幅降低了计算复杂度,使得高分辨率图像生成变得可行。

  2. 交叉注意力机制:通过交叉注意力机制将文本条件信息注入扩散过程,实现精确的文本到图像生成控制。

  3. 开源生态:作为开源模型,Stable Diffusion激发了大量的社区开发和创新应用,推动了文本到图像生成领域的快速发展。

  4. 潜在空间扩散:使用预训练 VAE 将图像压缩到潜在空间,在该空间进行扩散过程,大幅降低计算成本。

  5. 条件生成:通过交叉注意力机制将文本条件注入扩散过程,实现文本到图像的生成。

  6. 开源影响:Stable Diffusion 的开源发布推动了 AI 生成图像的民主化,催生了庞大的社区生态。

来源

相关